iT邦幫忙

ai agent相關文章
共有 297 則文章
鐵人賽 IT Operation DAY 13

技術 Day 13|最後一行是 Timeout,真正壞掉的地方卻在前面三層

自動化測試失敗時,畫面最後只留下了一行: TimeoutError: operation did not complete within 120 seconds...

鐵人賽 AI Security DAY 8

技術 Day 8|重試不是保險:Agent 如何把一個錯誤變成事故

Day 4 做完 timeout、退避重試和降級後,我本來以為這件事差不多收工了:SOP 查不到,最多重試幾次,然後不要開工單。 但那只限制了「同一個請求」。如...

鐵人賽 Claude AI DAY 23

技術 Day 23:把踩坑經驗回饋給 AI 工具本身——一個好的 bug report 長什麼樣

前言:這個問題該寫進 skill,還是該回報給工具本身? 「AI 又做了一件很奇怪的事,我要不要把這條規則寫進 CLAUDE.md,以後就不會再發生了?」 這個...

鐵人賽 AI Engineering DAY 23

技術 Day 23:架構決策的授權邊界——哪些決定不該讓 AI 自己拍板

前言:AI 判斷得出「這樣改比較好」,不代表它有資格決定要不要改 「AI 說這裡應該拆成兩個模組會比較好維護,那就照做啊,反正它講的技術理由也沒錯。」 這句話乍...

鐵人賽 Build on Google AI DAY 7

技術 [Day 6] 資料要活過隔天,先回答「這是誰的」

Part 3|第 7/30 篇 今日要做的事: 開好 Firebase 專案+Google 登入,讓「Verifier 已 ACCEPT 的餐點」能掛到固定 u...

鐵人賽 自我挑戰組 DAY 11

技術 11 環境變數地雷:launchd 找不到 nvm/node 怎麼辦

! 本篇文章將會介紹 環境變數地雷:launchd 找不到 nvm/node 怎麼辦,期望大家都能看懂 launchd 的精簡執行環境、學會診斷「手動會動、排程...

技術 模型在本機跑,不代表資料留在本機

GPU 裝在公司機房,inference server 也只開內網 IP。團隊鬆了一口氣,準備在簡報上寫「資料不出公司」。 但文件進模型之前,先被送到外部 em...

鐵人賽 AI Security DAY 7

技術 Day 7|Agent 不肯停下來:它能在幾分鐘內燒掉多少 Token?

Day 6 的 recursion_limit 解決了一件事:graph 不該無限繞圈。但我很快發現,step 數根本不能回答「這次到底花了多少」。一次 ste...

鐵人賽 Claude AI DAY 22

技術 Day 22:Code Review 也交給 AI——怎麼設計審查流程避免誤判

前言:讓 AI 審查 AI,是不是找了個裁判自己吹哨? 「讓另一個 AI agent 來 review 剛剛那個 AI agent 寫的程式碼,這樣真的有用嗎?...

鐵人賽 AI Engineering DAY 29

技術 Day 29|Agent 的權限可以做到哪一步:風險分級、人工確認與 Evals

Day 28 把 Rawdata 申請拆成五個 Tool。技術上,每個 Tool 都可以交給 Agent 呼叫;實際設計採分層授權,依動作逐步開放。 查詢資料表...

鐵人賽 IT Operation DAY 12

技術 Day 12|只改了三行 Code,摘要卻寫出了五個不存在的設計理由

一個小 Change 合併前,團隊請 AI 幫忙產生變更摘要。 Diff 很短。 大概只有幾行: - old routing condition + new r...

鐵人賽 Build on Google AI DAY 6

技術 [Day 5] 進庫前兩道閘門:壞了只救一次,看不懂就停

Part 2|第 6/30 篇 今日要做的事: 把餐點照接到「真的能寫進 today_meals」——結構壞了怎麼救、語意不穩怎麼問人。 今天要解決的目的: P...

鐵人賽 自我挑戰組 DAY 10

技術 10 寫第一個 launchd plist:排程 Hello World

! 本篇文章將會介紹 寫第一個 launchd plist:排程 Hello World,期望大家都能親手寫出第一份 plist、用 bootstrap 載入、...

鐵人賽 AI Engineering DAY 28

技術 Day 28|把服務藍圖變成工具:查規則、補資料、產生草稿、確認送出

Day 27 的目標很清楚:使用者說一次需求,Agent 先交出完成八成的申請草稿,使用者集中調整一次,再完成送出。 接下來要處理真正的技術問題。Agent 要...

鐵人賽 Claude AI DAY 21

技術 Day 21:多 Agent 協作——什麼情況該讓子任務跑在獨立 agent

前言:改動不大,是不是就不用委派? 「這個任務範圍很小,直接自己做不是比開一個獨立 agent 還快嗎?」 這是個很常見的直覺,而且這個直覺的判斷依據其實錯了。...

鐵人賽 自我挑戰組 DAY 0

技術 Day 06:跟 AI 一起規劃 30 天大綱時,人要保留哪些判斷

前言 「大綱都讓 AI 生成了,那還有什麼是需要人保留的?」 Day 02 講過大綱規劃的粗略分工:人定主題句跟邊界、AI 拆解結構。這篇要把「人保留的判斷」講...

鐵人賽 AI Security DAY 6

技術 Day 6|AI Agent 不是在思考,它其實是在不斷試錯

我一開始把 Agent 想得太像一個會「理解整個任務」的助手。實際把 Helpdesk Agent 拆開後,感覺比較像一個不停改變狀態的程式:模型看見目前資料,...

鐵人賽 IT Operation DAY 11

技術 Day 11|AI 查遍 Repository 說沒有,後來才發現問題根本沒問清楚

使用者問: 「有沒有可以 Reset Network 的功能?」 AI 開始 Search。 找到幾個很接近的東西: reset_adapter restart...

鐵人賽 AI 自動化 DAY 5

技術 Day 05|Hermes Agent Desktop 基本操作,及設定、切換 Agent 靈魂

前幾篇,我們完成了 Hermes Agent 的安裝與基本認識。 今天開始進入實際使用,首先我們先來認識 Hermes Desktop 的操作介面,接著設定 S...

鐵人賽 Build on Google AI DAY 5

技術 [Day 4] 餐點照終於進了 JSON,但模型突然不會說「不確定」

Part 2|第 5/30 篇 今日要做的事: 替餐點照定 MealAnalysisSchema,同一張鴨腿便當打開 Structured outputs 再跑...

鐵人賽 自我挑戰組 DAY 9

技術 09 為什麼是 launchd 而不是 cron:macOS 排程的正確姿勢

! 本篇文章將會介紹 為什麼是 launchd 而不是 cron:macOS 排程的正確姿勢,期望大家都能搞懂 macOS 排程的取捨邏輯,看懂 plist 每...

鐵人賽 AI Security DAY 5

技術 Day 5|我還沒讓 Agent 上線,先用 Promptfoo 打它一拳

前四天,我把這個練習專案拆得很保守:它只能查 mock SOP,然後在記憶體裡建立 mock 工單。 但程式能動,不代表我知道它會不會在改一行 prompt、補...

鐵人賽 AI Engineering DAY 27

技術 Day 27|從逐欄填表到一次確認:Agent 如何協助完成一張申請單

幫我申請某張業務資料表,每天抄寫一次,權限給資料分析團隊,最後交給王主管審核。 這是我想像中,第四代 DAP 的起點。 使用者先說明目的。Agent 取得資...

鐵人賽 Software Development DAY 11

技術 Day 11:讓 AI 遵守「先紅後綠再重構」的流程設計

前言 「我知道 TDD 的三個步驟,但要怎麼讓 AI 真的照著做,而不是嘴巴上說『好的,我會遵循 TDD』,實際上還是一次把東西全寫完?」 這是這幾天讀者留言裡...

鐵人賽 Claude AI DAY 20

技術 Day 20:記憶會過期——怎麼避免 AI 依賴已經失效的舊資訊

前言:AI 說「我記得」,是好事還是壞事? 「AI 有長期記憶,不用每次都重新解釋專案背景,這樣效率不是更高嗎?」 效率確實更高——直到那份記憶跟現實脫節的那一...

鐵人賽 IT Operation DAY 10

技術 Day 10|Repository 裡找得到,為什麼這台機器還是不能用?

一位工程師問 AI: 「這個操作有支援嗎?」 AI 搜 Repository。 很快找到一個名稱完全吻合的方法。 裡面甚至有完整參數和執行流程。 回答因此很乾脆...

鐵人賽 自我挑戰組 DAY 8

技術 08 Exit hooks:Agent 做完事自動觸發下一步

! 本篇文章將會介紹 Exit hooks:Agent 做完事自動觸發下一步,期望大家都能讓 agent 的生命周期自己開口說話,把「在外面等它做完」的苦差事交...

鐵人賽 Claude AI DAY 19

技術 Day 19:從「被使用者糾正」到「記住規則」——feedback 記憶怎麼運作

前言:記住「使用者不喜歡什麼」,真的有用嗎? 「AI 被糾正過的事情,記下來下次不要再犯不就好了嗎?」 聽起來理所當然,但真正動手設計這套記憶機制時,會發現「記...

鐵人賽 AI Security DAY 4

技術 Day 4|工具壞掉後,Agent 沒停下來,反而把問題越搞越大

工具失敗時,Agent 最危險的反應往往不是回覆錯誤,而是把同一個請求又送了一次。 Day 3 我只讓 Agent 查 mock SOP、建立 mock 工...

鐵人賽 AI Engineering DAY 26

技術 Day 26|第四代 DAP 的目標:讓 Agent 協助完成一張申請單

第四代 DAP 的使用方式,會從一句話開始: 幫我申請一張資料抄寫單。來源是某張業務資料表,每天更新,需要同步到雲端。 Agent 讀完後,先找到「資料抄寫...